<p>OpenAI के नवीनतम बिलिंग नियमों के अनुसार, GPT-5.6 Sol जैसे मॉडल अत्यधिक लंबे संदर्भ वाले अनुरोधों के लिए स्तरीय कीमतों का उपयोग करते हैं।</p><p>जब किसी एक अनुरोध का संदर्भ 272K tokens से अधिक हो जाता है, तो इनपुट, कैश रीड और आउटपुट की गणना उच्चतर स्तरीय कीमतों के आधार पर की जा सकती है। यह नियम OpenAI की आधिकारिक कीमतों से संबंधित है, AI-ROUTER द्वारा अस्थायी अतिरिक्त शुल्क या असामान्य बिलिंग नहीं है।</p><p></p><p>GPT-5.6 Sol की मानक कीमतों का उदाहरण:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> मद 272K तक 272K से अधिक</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> इनपुट $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> कैश रीड $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> आउटपुट $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>अंतिम शुल्क की गणना विशिष्ट समूह, खाते के गुणक और अन्य बिलिंग कॉन्फ़िगरेशन के आधार पर की जाएगी।</p><p></p><p>उपयोग रिकॉर्ड में दिखाई देने वाला x2 चिह्न बताता है कि इस अनुरोध पर लंबे संदर्भ की स्तरीय बिलिंग लागू हुई। यह चिह्न मुख्य रूप से यह दर्शाता है कि इनपुट/कैश रीड उच्चतर स्तर में चले गए हैं। इसका अर्थ यह नहीं है कि पूरे अनुरोध की सभी लागतें सीधे दोगुनी हो गई हैं; आउटपुट पर अलग स्तरीय गुणक लागू हो सकता है।</p><p></p><p><strong> ## स्तरीय बिलिंग लागू होने से कैसे बचें</strong></p><p>यदि आपको 1M Token संदर्भ विंडो की आवश्यकता नहीं है, तो Codex की संदर्भ सीमा को 272K के भीतर समायोजित करने की सलाह दी जाती है।</p><p></p><p>यह फ़ाइल खोलें:</p><p> ~/.codex/config.toml</p><p></p><p>लेख में दी गई मूल 1M कॉन्फ़िगरेशन:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>इसे बदलकर करें:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>सहेजने के बाद Codex को पुनः प्रारंभ करें और एक नया सत्र बनाएँ।</p><p></p><p>यदि आप इसे केवल किसी एक सत्र के लिए अस्थायी रूप से लागू करना चाहते हैं, तो यह कमांड उपयोग कर सकते हैं:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> साथ ही, यह सुझाव दिया जाता है:</p><p> - स्वचालित संक्षेपण समय पर सक्षम करें;</p><p> - अत्यधिक लंबे कार्यों को कई सत्रों में बाँटें;</p><p> - एक बार में लौटाए जाने वाले अत्यधिक मात्रा वाले टूल आउटपुट को कम करें;</p><p> - पुराने संवादों का नियमित रूप से सारांश बनाएँ और उन्हें साफ़ करें।</p><p></p><p>यदि आपको वास्तव में 1M Token संदर्भ विंडो की आवश्यकता है, तो आप मूल कॉन्फ़िगरेशन का उपयोग जारी रख सकते हैं, लेकिन 272K से अधिक होने पर OpenAI की उच्चतर स्तरीय कीमतों के अनुसार बिलिंग की जाएगी।</p><p></p><p>मूल कॉन्फ़िगरेशन की जानकारी के लिए देखें: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex में GPT-5.6 Sol के लिए 10 लाख Token संदर्भ विंडो कैसे सक्षम करें </a></p><p></p><p>आपकी समझ और समर्थन के लिए धन्यवाद।</p>